-
π₀.₇ 论文精读:用多模态提示把机器人基础模型变成可操控的通才精读 Physical Intelligence 的 π₀.₇:多模态 context、混合质量数据、子目标图像与异步 flow policy 如何带来灵巧、跨形态和组合泛化。
24 min read -
π₀.₅ 论文精读:面向开放世界泛化的 Vision-Language-Action 模型精读 π₀.₅:通过异构数据 co-training、层级 subtask 推理与 FAST/Flow 混合动作表示,让移动操作机器人在未见过的家庭环境中执行长时程整理任务。
30 min read -
π₀ 论文精读:通用机器人控制的视觉-语言-动作流模型精读 π₀:基于预训练 PaliGemma VLM 与 flow matching action expert,在 10000+ 小时跨形态机器人数据上预训练,并验证直接提示、语言指令和微调。
27 min read